메뉴

#음성 합성(TTS)

MP
MarkTechPost 34일 전
IMP 8

그래디움, GPT 모델 능가하는 실시간 음성 번역 모델 공개

AI 기업 그래디움이 20개 이상의 언어 쌍을 지원하는 실시간 음성 번역 모델인 stt-translate와 s2s-translate를 공개했습니다. 이 모델들은 기존의 복잡했던 3단계 처리 방식을 단순화하여 GPT 및 제미나이 실시간 번역 모델들을 뛰어넘는 정확도와 처리 속도(저지연)를 달성했습니다. 또한 사용자가 원하는 출력 음성을 선택하거나 복제(클로닝)할 수 있는 기능까지 지원하여 실시간 통역 및 번역 분야의 패러다임을 전환할 중요한 모델로 평가받습니다.

실시간 음성 번역 음성 인식(STT) 음성 합성(TTS)
LL
r/LocalLLaMA 76일 전
IMP 7

드라마박스: LTX 2.3 기반 역대 가장 풍부한 감정 표현 TTS

Resemble AI가 LTX 2.3을 기반으로 감정 표현이 지금까지 중 가장 뛰어난 음성 합성(TTS) 모델인 '드라마박스(DramaBox)'를 공개했습니다. 해당 모델은 깃허브(GitHub)와 허깅페이스(Hugging Face)에 오픈소스 및 데모 형태로 배포되어 개발자들이 즉시 테스트하고 활용할 수 있습니다.

음성 합성(TTS) 오픈소스 드라마박스